量子位
06-16 07:05
4步出声,单卡0.24秒!Noiz AI联合港科大清华,开源音频生成大模型
📌 一句话:国产AI音频模型实现"出生"速度突破,单卡0.24秒即可生成,刷新行业纪录。
💡 3个要点
速度革命:单卡仅需0.24秒完成音频生成,比主流模型快数十倍
顶尖联合:Noiz AI与港科大、清华共同研发,完全开源可免费商用
极简架构:仅需4步迭代即可出声,大幅降低算力门槛
📖 背景
此前音频生成大模型普遍面临生成慢、算力成本高的痛点,Suno等国际产品的生成等待时间成为用户体验瓶颈。
💭 点评
开源音频生成模型的意义不亚于当年LLaMA对大语言模型的推动。当技术门槛从"烧钱"变成"人人可用",真正的应用爆发才会到来。速度的背后是工程实力的体现,也是国产AI在全球竞争中的硬气底牌。 ---
📡 来源:量子位
📖 原文链接
点击阅读原文 →